用3D几何先验驱动视频扩散,实现更一致的世界生成
用3D几何先验驱动视频扩散,实现更一致的世界生成随着视频扩散模型能力不断提升,从单张图像出发、按照用户指定的相机轨迹生成新视角视频,正在成为 World Modeling 的重要技术路线。
搜索
随着视频扩散模型能力不断提升,从单张图像出发、按照用户指定的相机轨迹生成新视角视频,正在成为 World Modeling 的重要技术路线。
图像生成模型正从「会创作」转向「可操作」。
该项目名为 Anatomy Atelier,是一款面向人体解剖学习的交互式 3D 网页应用。它把器官模型、知识卡片和交互操作放在同一个界面,我们通过旋转、缩放和点击,更直观地理解人体结构。
从 2D 像素到 3D 场景 Query,影溯正在尝试把三维内容生产推向可规模化调用的新阶段。
如何从一段视频中获得完整、稳定的 3D 物体?过去,这个问题大致沿着两条路线发展。
近日,比特无限发布的 Arko-T,是一款面向 Text-to-Structured 3D Generation 的 4B 参数基础模型。该模型由比特无限联创、首席科学家周平义博士带队完成。它接收自然语言描述,直接输出可执行的 Build123d 程序。程序经过 CAD 内核运行后,可以得到带有命名参数、结构特征和建模过程的 CAD 设计实体。
3D打印无疑是全球增长最受关注的赛道之一,但结构化、可编辑的物理3D数据却极度稀缺。就在这个行业真空里,一家年轻公司浮出水面——AI生成矢量3D模型的比特无限(BitInf)。
近日,来自清华大学等单位的研究团队提出了AutoMIA,一种自动生成镜像错觉艺术的 AI 设计方法,用户仅需任意指定两张图片,分别对应镜子前和镜子中的图案,AutoMIA就可以自动完成3维艺术品的设计,并且支持直接3D打印出来制作艺术品。
国防科技大学虚拟现实与视觉计算团队(SAW Lab)联合先进制导与控制技术国家级重点实验室等推出面向航拍几何 3D 视觉的统一大规模数据集与评测基准 「AirZoo」。
7 月 20 日,Meshy 宣布完成近 4 亿美元 B 轮融资,投后估值超过 100 亿元人民币。这是它成立以来第一次对外公布估值,一出手就刷新了 AI 3D 赛道单轮融资规模与估值两项纪录。据公司披露,这也是全球 AI 3D 领域迄今最高的一个估值。